对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回
对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回AgnesCode在部分芯片上跑出更高性能,免费模型完成专业级交付。
搜索
AgnesCode在部分芯片上跑出更高性能,免费模型完成专业级交付。
OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
文章拆解了 Astra 模型与 Codex Harness 的配合方式:Codex 启动一个持续运行的代码环境,接入浏览器和桌面操作工具;Astra 通过无障碍模式读取界面中的文字、按钮结构,并通过截图综合判断。模型把准备执行的操作写成代码,交给 Codex 的工具完成。
OpenAI Codex团队成员Eric Provencher发文建议用户尽快清理项目中的Skill文件、AGENTS.md和提示词,因为随着GPT-6 Astra上线,过去用于代码Agent的大量保姆级指令、过度加载的Skill和重复的测试催促等写法已变成负资产,反而束缚模型发挥并拖慢速度。
Superdesign 近日在 Codex(ChatGPT)插件市场上线官方插件,可让 Codex 自动扫描项目设计资产并在右侧画布流式渲染 UI,Agent 还会自检迭代,用户选定后一键将设计代码应用回本地项目。
就在刚刚,GPT-6 Astra 毫无预警地全量上线。GPT-6 Astra 已经正式面向 ChatGPT Work 以及 Codex 的 Pro、Enterprise 和 Business Premium 用户同步开放,API 接口也已经全部就绪。
前DeepMind AI Scientist团队创立的Inherent获5000万美元种子融资,其基于Qwen3.6-27B后训练的科研判断系统Faraday在AI for Science预留测试集上以0.791的平均得分超越Claude Opus 4.8与GPT-5.5 Codex。
趁着这个重置额度,做了几个小工具,今天要分享的就是其中一个。一个 Codex 桥接 ChatGPT 的 SKILL 技能,开源了。5.6 Sol 很强,在 Codex 桌面端拿它处理复杂任务,额度消耗得很快,特别是 Codex Plus 用户,已经恢复了5小时的窗口限制,稍微写一个复杂的技术方案,可能问几个问题,5小时的额度就干没了,这种体验很差。
8 月 26 日,群核科技正式发布了 AI 3D 生成模型 Lux3D。它提供标准版、极速版和渲染器能力,还能通过 API、插件接入 Codex、WorkBuddy 等 Agent 及主流设计工作流。
这个周末,Coding Agent 用户同时看到了两种截然不同的「额度调整」。一边,Codex 负责人 Tibo(Thibault Sottiaux)再次按下了那个已经快被用户玩成梗的「重置按钮」:所有 Codex 和 ChatGPT Work 付费用户的使用额度,将获得一次重置。